
Anthropic 的 Claude AI 模型在導入隱形「AI浮水印」後,市面上迅速出現多款聲稱能移除浮水印的工具,引發內容驗證與AI倫理的討論。
美國人工智慧公司 Anthropic 近日更新其大型語言模型 Claude,於生成的內容中嵌入「AI浮水印(Watermark)」(一種隱藏的數位標記,用於識別內容是否由AI生成)。此舉不僅在AI產業引起關注,更在數日內迅速催生了AI浮水印移除工具的市場,顯示出對AI內容驗證技術的攻防戰正快速升溫。
根據《SC Media》報導,Anthropic 實施這項措施後,網路上隨即出現多款旨在消除 AI 浮水印的工具,包括在程式碼代管平台 GitHub 上一個名為「watermarks-remover」的專案,已獲得逾 4,500 個星號(意指該專案受到開發者廣泛關注與肯定)。其他如「claude-watermark-cleaner」和「remove-ai-watermarks」等工具也相繼問世。部分服務甚至宣稱能支援 OpenAI 和 Google 旗下 Gemini 模型所生成的浮水印內容。
報導指出,這些新興工具的技術細節多數集中於去除內容中的「中繼資料(Metadata)」或隱藏字元。這類移除方式相對不複雜。然而,Anthropic 埋入的 AI 浮水印實際上是透過 AI 模型在文字選擇上的細微模式來實現,而非簡單的附加資料。若要徹底移除此類浮水印,將需要大幅度改寫文本內容,才能改變其底層的語言模式。開發者 Guillaume Meyer 也坦言,他開發的工具「watermarks-remover」尚未具備實際移除浮水印的功能。
這波浮水印移除工具的出現,突顯了 AI 內容供應鏈中潛在的風險。在 Anthropic 尚未公開其浮水印檢測方法的情況下,驗證移除工具的成效極具挑戰性。此現象也讓外界對於 AI 生成內容的真偽驗證更加擔憂,尤其是在《歐盟人工智能法案》等法規強調 AI 透明度的背景下,如何確保數位內容的真實性,將是未來 AI 發展的重要課題。
